Top

Log Dosyası Analizine Sıfırdan Başlamak: Araçlar ve İlk 30 Dakika

Log Dosyası Analizine Sıfırdan Başlamak: Araçlar ve İlk 30 Dakika - kapak görseli

Log Dosyası Analizine Sıfırdan Başlamak: Araçlar ve İlk 30 Dakika

Log dosyası analizi, teknik SEO’da herkesin değerini kabul ettiği ama çok az kişinin gerçekten yaptığı iş. Sebep genelde konuyu bilmemek değil; dosyaya nasıl ulaşılacağını, hangi aracın açılacağını ve ilk olarak neye bakılacağını bilmemek.

Bu yazı tam olarak o boşluğu doldurmak için. Log verisinin yapay zekâ görünürlüğü açısından ne anlattığını daha önce Log Dosyaları: AI Arama Stratejisinin Görmezden Gelinen Verisi yazısında ele almıştım; burada ise işin mutfak kısmı var. Diğer teknik içerikler için ana sayfayı takip edebilirsiniz.

İçindekiler

Log Dosyası Analizine Sıfırdan Başlamak: Araçlar ve İlk 30 Dakika yol haritası

Log Dosyasına Nasıl Erişilir?

Erişim, işin en çok takılınan adımı — ve çoğu zaman gerçekte olduğundan daha zor sanılıyor.

Paylaşımlı hosting kullanıyorsanız, panelde genellikle “Ham Erişim Kayıtları” ya da “Raw Access Logs” adında bir bölüm var. Varsayılan olarak kapalı gelebiliyor; açtığınızda sıkıştırılmış günlük dosyalar birikmeye başlıyor. Panelde göremiyorsanız destek ekibine sormak yeterli, çoğu sağlayıcı talep üzerine açıyor.

Kendi sunucunuz varsa dosyalar zaten yerinde: Apache için genelde /var/log/apache2/access.log, Nginx için /var/log/nginx/access.log yolunda duruyor. Burada dikkat edilecek tek şey, log döndürme ayarının kaç günlük veriyi sakladığı.

Önünüzde bir CDN varsa durum biraz değişiyor: bu durumda ziyaretçilerin çoğu sunucunuza hiç ulaşmadığı için sunucu logu eksik kalıyor. Doğru kaynak CDN sağlayıcısının kendi log dışa aktarma özelliği oluyor; bu özellik genelde daha üst paketlerde açılıyor.

Bir de dosya formatı meselesi var. Standart birleşik log formatında her satır sırayla IP, zaman damgası, istek satırı, durum kodu, boyut, referans ve kullanıcı aracısı içeriyor. Bu alanların hepsine ihtiyacınız yok; SEO analizi için üçü yeterli: istenen URL, durum kodu ve kullanıcı aracısı.

Hangi Ölçekte Hangi Araç?

Araç seçiminde belirleyici olan sitenin sayfa sayısı ve log dosyasının boyutu.

Birkaç bin sayfaya kadar: Elektronik tablo yeterli. Dosyayı sütunlara ayırıp filtre uygulamak, pivot tabloyla URL bazında saydırmak — hepsi klasik tablo işlemleri. Milyonlarca satırda tablo programları tıkanıyor ama orta ölçekte tamamen iş görüyor.

Orta ve büyük siteler: Screaming Frog’un log analiz aracı bu iş için tasarlanmış; tarama verisiyle log verisini birleştirip “taranmayan sayfalar” gibi listeleri doğrudan çıkarabiliyor. Semrush’ın log aracı da benzer işi görüyor ve mevcut SEO panelinizle entegre çalışıyor.

Tekrarlayan analiz gerekiyorsa: Python en esnek yol. Birkaç satırlık bir betikle her ay aynı raporu üretebiliyorsunuz. İskelet şu kadar basit:

import re, collections
bot = re.compile(r"Googlebot|GPTBot|PerplexityBot|ClaudeBot")
sayac = collections.Counter()
with open("access.log", encoding="utf-8", errors="ignore") as f:
    for satir in f:
        if not bot.search(satir):
            continue
        parca = satir.split('"')
        url = parca[1].split(" ")[1] if len(parca) > 1 else ""
        sayac[url] += 1
for url, adet in sayac.most_common(30):
    print(adet, url)

Bu betik, bot isteklerini URL bazında sayıp en çok taranan otuz sayfayı listeliyor. İlk analiz için fazlasıyla yeterli.

İlk 30 Dakikada Yapılacak Analiz

İlk oturumda her şeyi anlamaya çalışmayın. Dört soruya cevap arayın, yeter.

Birinci soru: Hangi botlar geliyor ve hangi oranda? Kullanıcı aracısı alanına göre gruplayıp saydırın. Googlebot’un payı beklendiği gibi mi, yapay zekâ tarayıcılarının payı ne durumda? Bu tek tablo bile çoğu ekipte sürpriz yaratıyor.

İkinci soru: En çok taranan yirmi sayfa hangileri? Bu liste, arama motorlarının sitenizi nasıl gördüğünü gösteriyor. Listede en değerli içerikleriniz yoksa, iç link yapınızda ya da site haritanızda bir sorun var demektir.

Üçüncü soru: Hangi sayfalar hiç taranmıyor? Bunu bulmak için site haritanızdaki URL listesiyle logdaki URL listesini karşılaştırın; aradaki fark, arama motorlarının hiç uğramadığı sayfalar. Search Console’daki “keşfedildi ama indekslenmedi” uyarısının cevabı genelde tam burada saklı.

Dördüncü soru: Botlar hangi durum kodlarını alıyor? Bot isteklerinin içinde 4xx ve 5xx oranı yüksekse, tarama kapasitesinin bir kısmı boşa gidiyor demektir. 404’lerin hangisine müdahale etmek gerektiğini 404 taraması üzerine yazdığım yazıda ayrıntılı ele aldım.

Bu dört sorunun cevabını bir tabloya yazıp saklayın. Değeri, tek seferlik fotoğraftan çok aylar içindeki değişimde ortaya çıkıyor.

Log Verisinin En Çok İşe Yaradığı Üç Senaryo

Site taşıma sonrası kontrol. Yeni yapıya geçtikten sonra botların eski URL’lere gitmeye devam edip etmediğini, yönlendirmelerin doğru çalışıp çalışmadığını gerçek zamanlı görebiliyorsunuz. Search Console’un raporu günler sonra güncellenirken log verisi ertesi gün elinizde.

Büyük katalog sitelerinde tarama israfı. Filtre kombinasyonlarından doğan sonsuz URL’ler, e-ticaret sitelerinde tarama kapasitesinin ciddi bir kısmını yutabiliyor. Bu israfın gerçekten var olup olmadığını yalnızca log verisi kanıtlıyor; varsayımla robots kuralı yazmak çoğu zaman işe yarayan sayfaları da kapatıyor.

Yeni içeriğin keşfedilme süresi. Yayınladığınız bir yazının kaç gün sonra ilk kez tarandığını ölçmek, iç linkleme ve site haritası çalışmalarınızın gerçekten işe yarayıp yaramadığını gösteren en dolaysız metrik. Bu süre haftalarla ifade ediliyorsa, keşfedilebilirlik tarafında yapısal bir sorununuz var.

Saklama Süresi ve KVKK Tarafı

Log dosyaları IP adresi içeriyor ve IP adresi Türkiye mevzuatında kişisel veri sayılabiliyor. Bu, log tutmanın yasak olduğu anlamına gelmiyor — güvenlik ve sistem yönetimi için tutulması meşru bir amaç. Ama iki şeye dikkat etmek gerekiyor.

Birincisi saklama süresi. Belirsiz süreyle saklamak yerine bir süre belirleyip buna uymak doğru yaklaşım; SEO analizi için üç ay çoğu ihtiyacı karşılıyor, altı ay ise mevsimsel karşılaştırma yapmaya imkân veriyor. İkincisi aydınlatma metniniz: sunucu kayıtlarının tutulduğunu, hangi amaçla ve ne kadar süreyle saklandığını gizlilik politikanızda belirtmek gerekiyor.

Analizi bir üçüncü tarafa ya da bulut aracına yaptırıyorsanız, IP alanını analiz öncesinde maskelemek hem yasal riski hem gereksiz veri paylaşımını azaltıyor — SEO analizi için IP’ye zaten ihtiyacınız yok.

Diğer teknik yazılar için SEO kategorisine göz atabilirsiniz.

Sıkça Sorulan Sorular

Hosting sağlayıcım log vermiyor, alternatif var mı?

Sunucu tarafında hafif bir kayıt katmanı kurmak ya da CDN log dışa aktarma özelliğini kullanmak iki alternatif. Hiçbiri mümkün değilse Search Console’un tarama istatistikleri raporu kısmi bir görüntü veriyor — sayfa bazında detay yok ama genel eğilim görülebiliyor.

Kullanıcı aracısı taklit edilebiliyor, veri güvenilir mi?

Sahte Googlebot iddiaları gerçekten oluyor. Kritik analizlerde IP adresini ters DNS sorgusuyla doğrulamak gerekiyor; Google bu doğrulama için resmi IP aralıklarını yayımlıyor. Genel eğilim analizinde bu adımı atlamak sorun yaratmıyor, ama “botlar sitemi eziyor” gibi bir sonuca varmadan önce doğrulama şart.

Ne sıklıkla analiz yapmalıyım?

Ayda bir yeterli. Site taşıma, büyük yapı değişikliği ya da ani trafik düşüşü gibi durumlarda ise haftalık bakmak mantıklı. Günlük takip, çok büyük siteler dışında getirdiğinden fazla zaman alıyor.

Küçük sitede zahmete değer mi?

Küçük sitede analiz daha kolay ve bulgular daha nettir. Yüz sayfalık bir sitede on sayfanın hiç taranmadığını görmek, o on sayfayı aynı gün düzeltmek anlamına geliyor. Zaman maliyeti de düşük — dosya küçük olduğu için tablo programı fazlasıyla yetiyor.

Log analizi Search Console’un yerini tutar mı?

İkisi farklı şeyler söylüyor. Search Console size Google’ın kararlarını gösteriyor: neyi indeksledi, neyi almadı. Log ise ham davranışı gösteriyor: gerçekte nereye geldi, ne aldı. Sorunun nedenini bulmak için genelde ikisine birlikte bakmak gerekiyor.

Aklınızda Kalsın

Log analizi bilgi meselesinden çok alışkanlık meselesi. Bir kez erişimi kurup betiği yazdığınızda, sonraki her ay yarım saatlik bir işe dönüşüyor.

Bu hafta yapılacak iş net: hosting panelinizi açın, ham erişim kayıtlarının açık olup olmadığını kontrol edin. Kapalıysa açın; açıksa son yedi günün dosyasını indirip yukarıdaki dört soruyu cevaplayın. Çıkan tablo, muhtemelen sitenizin nasıl tarandığına dair bugüne kadarki varsayımlarınızın bir kısmını değiştirecek.

Teknik denetim tarafında destek isterseniz SEO & SEM danışmanlığı sayfasından iletişime geçebilirsiniz.

Kaynakça

Search Engine Journal. (2026). Ask an SEO: Should SEOs use log file data? https://www.searchenginejournal.com/ask-an-seo-should-seos-use-log-file-data/567932/

Content Marketing Institute. (2026, Mart). Try this underused tactic to get your content cited in AI search. https://contentmarketinginstitute.com/generative-engine-optimization/content-cited-in-ai-search


Hasan Yasin TÜRKYILMAZ sitesinden daha fazla şey keşfedin

Subscribe to get the latest posts sent to your email.

No Comments